Skip to content
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>OpenAI के नवीनतम बिलिंग नियमों के अनुसार, GPT-5.6 Sol जैसे मॉडल अत्यधिक लंबे संदर्भ वाले अनुरोधों के लिए स्तरीय कीमतों का उपयोग करते हैं।</p><p>जब किसी एक अनुरोध का संदर्भ 272K tokens से अधिक हो जाता है, तो इनपुट, कैश रीड और आउटपुट की गणना उच्चतर स्तरीय कीमतों के आधार पर की जा सकती है। यह नियम OpenAI की आधिकारिक कीमतों से संबंधित है, AI-ROUTER द्वारा अस्थायी अतिरिक्त शुल्क या असामान्य बिलिंग नहीं है।</p><p></p><p>GPT-5.6 Sol की मानक कीमतों का उदाहरण:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> मद 272K तक 272K से अधिक</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> इनपुट $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> कैश रीड $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> आउटपुट $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>अंतिम शुल्क की गणना विशिष्ट समूह, खाते के गुणक और अन्य बिलिंग कॉन्फ़िगरेशन के आधार पर की जाएगी।</p><p></p><p>उपयोग रिकॉर्ड में दिखाई देने वाला x2 चिह्न बताता है कि इस अनुरोध पर लंबे संदर्भ की स्तरीय बिलिंग लागू हुई। यह चिह्न मुख्य रूप से यह दर्शाता है कि इनपुट/कैश रीड उच्चतर स्तर में चले गए हैं। इसका अर्थ यह नहीं है कि पूरे अनुरोध की सभी लागतें सीधे दोगुनी हो गई हैं; आउटपुट पर अलग स्तरीय गुणक लागू हो सकता है।</p><p></p><p><strong> ## स्तरीय बिलिंग लागू होने से कैसे बचें</strong></p><p>यदि आपको 1M Token संदर्भ विंडो की आवश्यकता नहीं है, तो Codex की संदर्भ सीमा को 272K के भीतर समायोजित करने की सलाह दी जाती है।</p><p></p><p>यह फ़ाइल खोलें:</p><p> ~/.codex/config.toml</p><p></p><p>लेख में दी गई मूल 1M कॉन्फ़िगरेशन:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>इसे बदलकर करें:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>सहेजने के बाद Codex को पुनः प्रारंभ करें और एक नया सत्र बनाएँ।</p><p></p><p>यदि आप इसे केवल किसी एक सत्र के लिए अस्थायी रूप से लागू करना चाहते हैं, तो यह कमांड उपयोग कर सकते हैं:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> साथ ही, यह सुझाव दिया जाता है:</p><p> - स्वचालित संक्षेपण समय पर सक्षम करें;</p><p> - अत्यधिक लंबे कार्यों को कई सत्रों में बाँटें;</p><p> - एक बार में लौटाए जाने वाले अत्यधिक मात्रा वाले टूल आउटपुट को कम करें;</p><p> - पुराने संवादों का नियमित रूप से सारांश बनाएँ और उन्हें साफ़ करें।</p><p></p><p>यदि आपको वास्तव में 1M Token संदर्भ विंडो की आवश्यकता है, तो आप मूल कॉन्फ़िगरेशन का उपयोग जारी रख सकते हैं, लेकिन 272K से अधिक होने पर OpenAI की उच्चतर स्तरीय कीमतों के अनुसार बिलिंग की जाएगी।</p><p></p><p>मूल कॉन्फ़िगरेशन की जानकारी के लिए देखें: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex में GPT-5.6 Sol के लिए 10 लाख Token संदर्भ विंडो कैसे सक्षम करें </a></p><p></p><p>आपकी समझ और समर्थन के लिए धन्यवाद।</p>
  • 0 Votes
    1 Posts
    69 Views
    A
    <p>OpenAI के नवीनतम बिलिंग नियमों के अनुसार, GPT-5.6 Sol जैसे मॉडल अत्यधिक लंबे संदर्भ वाले अनुरोधों के लिए स्तरीय कीमतों का उपयोग करते हैं।</p><p>जब किसी अनुरोध का संदर्भ 272K tokens से अधिक हो जाता है, तो इनपुट, कैश रीड और आउटपुट की गणना ऊंची स्तरीय कीमतों के आधार पर की जा सकती है। यह नियम OpenAI की आधिकारिक कीमतों से संबंधित है, AI-ROUTER द्वारा अस्थायी अतिरिक्त शुल्क या असामान्य कटौती नहीं है।</p><p></p><p>GPT-5.6 Sol की मानक कीमतों का उदाहरण:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> मद 272K तक 272K से अधिक</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> इनपुट $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> कैश रीड $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> आउटपुट $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>अंतिम शुल्क की गणना अब भी विशिष्ट समूह, खाते के गुणक और अन्य बिलिंग कॉन्फ़िगरेशन के आधार पर की जाएगी।</p><p></p><p>उपयोग रिकॉर्ड में दिखाई देने वाला x2 चिह्न बताता है कि इस अनुरोध पर लंबे संदर्भ वाली स्तरीय बिलिंग लागू हुई। यह चिह्न मुख्य रूप से यह दर्शाता है कि इनपुट या कैश रीड ऊंचे स्तर में चले गए हैं; इसका अर्थ यह नहीं है कि पूरे अनुरोध के सभी शुल्क साधारण रूप से दोगुने हो गए हैं। आउटपुट पर अलग स्तरीय गुणक लागू हो सकता है।</p><p></p><p><strong> ## स्तरीय बिलिंग लागू होने से कैसे बचें</strong></p><p>यदि आपको 1M Token संदर्भ विंडो की आवश्यकता नहीं है, तो Codex की संदर्भ सीमा को 272K के भीतर वापस समायोजित करने की सलाह दी जाती है।</p><p></p><p>यह फ़ाइल खोलें:</p><p> ~/.codex/config.toml</p><p></p><p>मूल लेख में दी गई 1M कॉन्फ़िगरेशन:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>इसे इस प्रकार बदलें:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>सहेजने के बाद Codex को पुनरारंभ करें और नया सत्र शुरू करें।</p><p></p><p>यदि आप इसे केवल किसी एक सत्र के लिए अस्थायी रूप से लागू करना चाहते हैं, तो यह कमांड इस्तेमाल कर सकते हैं:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> साथ ही, यह सुझाव दिया जाता है:</p><p> - समय पर स्वचालित संक्षेपण सक्षम करें;</p><p> - अत्यधिक लंबे कार्यों को कई सत्रों में विभाजित करें;</p><p> - एक बार में लौटाए जाने वाले बड़े टूल आउटपुट को कम करें;</p><p> - पुराने संवाद की सामग्री का नियमित रूप से सारांश बनाकर उसे साफ़ करें।</p><p></p><p>यदि आपको वास्तव में 1M Token संदर्भ विंडो की आवश्यकता है, तो आप मूल कॉन्फ़िगरेशन का उपयोग जारी रख सकते हैं। हालांकि, 272K से अधिक होने पर OpenAI की ऊंची स्तरीय कीमतों के अनुसार शुल्क लिया जाएगा।</p><p></p><p>मूल कॉन्फ़िगरेशन संबंधी जानकारी के लिए देखें: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex में GPT-5.6 Sol के लिए 1 मिलियन Token संदर्भ विंडो कैसे सक्षम करें </a></p><p></p><p>आपकी समझ और समर्थन के लिए धन्यवाद।</p>